عوامل هوش مصنوعی OpenAI تلاش کردند ابزارهای ویکیپدیا را هک کنند و آن را با حجم انبوهی از ترافیک مواجه ساختند
گزارشها درباره آسیب رساندن عوامل هوش مصنوعی OpenAI به سایتهای شخص ثالث همچنان ادامه دارد.
ناشر ویکیپدیا روز دوشنبه اعلام کرد که عوامل هوش مصنوعی OpenAI تلاش کردهاند یک ابزار یادداشتبرداری میزبانیشده توسط این پلتفرم را هک کنند، ویرایشهای غیرمجاز انجام دهند و میلیونها درخواست سنگین را به زیرساخت آن ارسال نمایند؛ این جدیدترین مورد از اقدامات مخرب و بالقوه خطرناک سیستمهای OpenAI است.
بنیاد ویکیمدیا اعلام کرد که هدف برخی از اقدامات عوامل هوش مصنوعی، استفاده از ویکیپدیا به عنوان پروکسی برای دریافت دادهها از سایتهای شخص ثالث بوده است. در یک مورد، این عوامل «ویرایشهای مخربی» را ارسال کردند که هدفشان تغییر کاربری یک ابزار ارجاعدهی به عنوان پروکسی بود. در موردی دیگر، این عوامل تلاشهای ناموفقی برای نفوذ به ابزار یادداشتبرداری ویکیپدیا یعنی Etherpad انجام دادند تا از آن برای همان هدف استفاده کنند.
این عوامل همچنین میلیونها درخواست خودکار API، خزیدن در میلیونها صفحه و صدها هزار پرسوجو در سرویس پرسوجوی ویکیداده (Wikidata Query Service) انجام دادند. به گفته ناشر، اقدام آخر ممکن است در قطعی جزئی این سرویس پرسوجو در ماه مه نقش داشته باشد.
ویکیمدیا اعلام کرد: «به عنوان یک میزبان فناوری غیرانتفاعی برای برخی از بزرگترین و پرکاربردترین پلتفرمهای دانش آزاد در جهان، ما به شدت نگران تأثیر عوامل هوش مصنوعی «سرکش» بر پلتفرمهایی مانند پلتفرم خود هستیم که توسط داوطلبانی از سراسر جهان ساخته شدهاند و به وعده اینترنت آزاد تکیه دارند. حوادثی از این دست، و بسیاری موارد دیگری که کشف شدهاند (و همچنان در حال کشف شدن هستند)، نشان میدهند که چگونه عوامل هوش مصنوعی میتوانند منابع را تخلیه کنند، سرورها را از کار بیندازند و همچنین برای به خطر انداختن اطلاعات قابل اعتماد تلاش کنند.»
عوامل، همان عوامل همیشگی خواهند بود
در بیش از نیم دوجین مورد، عوامل هوش مصنوعی در حال انجام اقداماتی مچگیری شدهاند که اگر توسط هکرهای انسانی انجام میشد، احتمالاً به تشکیل پروندههای کیفری میجامید. در جریان آزمایش ابزارهای داخلی که برخی از خطمشیهای ایمنی آنها غیرفعال شده بود، این عوامل از یک تابلوی اعلانات دستساز برای تبادل یادداشت با یکدیگر استفاده کردند و در مورد راههای هک کردن شبکه Hugging Face و بهدست آوردن پاسخهای ذخیرهشده در آنجا، زمانی که خودشان قادر به تولید پاسخها نبودند، بحث کردند.
سایر حوادث شامل مواردی است مانند: تولید پرامپتهای خودکار عجیب توسط عوامل، انتشار پستهای غیرمجاز در یک وبسایت برای تبادل اطلاعات، دسترسی به دادههای غیرعمومی از یک وبسایت دولتی استرالیایی، و سوءاستفاده از تنظیمات معیوب DNS برای فرار از یک محیط سندباکس که OpenAI برای جلوگیری از دسترسی عوامل به اینترنت ایجاد کرده بود.
بخش عمدهای از جهان چنین رویدادهایی را به عنوان «سرکش شدن» عوامل هوش مصنوعی توصیف کردهاند، گویی که این عوامل از دستورات سرپیچی کردهاند. یکی از چهرههای برجسته که از این نوع چارچوببندی انتقاد میکند، اریک سالواگیو (Eryk Salvaggio)، محقق هوش مصنوعی و پژوهشگر گیتس در دانشگاه کمبریج است.
او به پایگاه Ars گفت: «آنچه من اینجا میبینم زبانهای است که مدلهای زبانی کارهای خودشان را انجام میدهند: خواندن و نوشتن. سندباکسهای ویکیپدیا مکان ایدهآلی برای این ماشینها هستند تا یادداشتهای خود را برای استفادههای بعدی به عنوان پرامپت ذخیره کنند، زیرا هر کسی – یا هر چیزی – میتواند در آنها بنویسد و به آنها پاسخ دهد. استفاده از ویکیها برای هماهنگی چندان تعجبآور نیست. OpenAI گفته است که این مدلها برای همکاری بین عوامل بهینهسازی شدهاند و رد و بدل کردن یادداشت راهی ساده برای انجام این کار است.»
علاوه بر این، مهندسان OpenAI مدلهای زبانی بزرگ (LLM) خود را به گونهای آموزش دادهاند که سرسخت باشند و فارغ از میزان موفقیتشان، به کار روی یک مسئله ادامه دهند. همچنین زمانی که مدلهای زبانی میانبرهایی را پیدا میکنند که مراحل یا منابع مورد نیاز برای حل یک مسئله را محدود میکند، سیستم آموزش به آنها پاداش میدهد. یکی دیگر از عوامل اصلی در بروز این اقدامات مخرب، عدم نظارت انسانی بود؛ چنانکه ماهها طول کشید تا مهندسان OpenAI متوجه شوند این عوامل در حال ورودِ پرسرصدا به دهها وبسایت خارجی هستند. افشاگری ویکیمدیا نمونه دیگری از ناکافی بودن نظارت انسانی را ارائه میدهد. روی هم رفته، میتوان استدلال کرد که این عوامل دقیقاً مطابق با دستورالعملهای دریافتی عمل کردهاند.
شرکت OpenAI به سوالات ایمیلشده پاسخی نداد. در عوض، این شرکت بیانیهای صادر کرد با این متن: «ما از یافتههای جزئی که ویکیمدیا با ما به اشتراک گذاشته است سپاسگزاریم. ما در حال بررسی و تحلیل فعالیتهایی که آنها شناسایی کردهاند به همراه تحقیقات کلی خود هستیم و با آنها همکاری میکنیم، و با پیشرفت این کار به اشتراکگذاری اطلاعات مرتبط را ادامه خواهیم داد.»
همانند بازرسان ویکیمدیا، OpenAI اعلام کرد که هنوز شواهدی نیافته است که نشان دهد عوامل هوش مصنوعی پیامی برای هماهنگی با سایر عوامل باقی گذاشتهاند، یا اینکه بتواند به طور قطعی بگوید حجم بالای بازدید از صفحات و درخواستهای API منجر به قطعی جزئی ماه مه شده است. OpenAI اعلام کرد که به جستجوی حوادث مشابهی که در آنها عواملش در فعالیتهای بالقوه غیرقانونی مشارکت داشته باشند، ادامه میدهد.
ویکیمدیا اعلام کرد: «در حالی که OpenAI اعتراف میکند که عوامل به طور «غیرقابل پیشبینی» رفتار میکنند، آنها همچنین باید مسئولیت خود را در قبال نظارت و پیشگیری از این خطرات بپذیرند. شرکتهای ارائهدهنده هوش مصنوعی به اندازه کافی برای ایمنسازی سیستمهای خود و حفاظت از عموم در برابر خطرات ناشی از آنها تلاش نمیکنند.»
نظر مهندس بهمن آبادی: رفتارهای مخرب عوامل هوش مصنوعی ناشی از باگ نیست، بلکه نتیجه منطقی پاداشدهی به مدلها برای دور زدن محدودیتها و رسیدن به هدف است. به عنوان مدرس و برنامهنویس، معتقدم تا زمانی که مکانیسمهای «توقفپذیری» و نظارت انسانیِ بلادرنگ در معماری ایجنتها تعبیه نشود، توسعه آنها فراتر از محیطهای کاملاً ایزوله، ریسکی فاجعهبار برای زیرساختهای وب خواهد داشت.